第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol
第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 SolKimi K3 发布十天后,AI 原生云服务商 Together AI 公布了一份独立评测报告。
来自主题: AI产品测评
9199 点击 2026-08-10 15:06
搜索
Kimi K3 发布十天后,AI 原生云服务商 Together AI 公布了一份独立评测报告。
发布之前,我在 X 上看到有人说,测 K3 的感觉就像在测 Fable 5。虽然离 Fable 5 还差一点点 🤏,但超过 Opus 4.8 和 GPT 5.5 基本没有问题。在前端能力,K3 的提升非常明显,我已经用它复刻了前段时间爆火的独立工作室 Abeto 推出的一款 3D 网页游戏 《 Messenger》(ps. 音乐手动配的,主角模型是 K3 自己判断、自主去游戏官网找的)
今天凌晨看到 Arena AI 更新 Code Arena 榜单时,我第一反应是有点意外。刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。